iT邦幫忙

2026 iThome 鐵人賽

DAY 30
0

前情

Day 29 把這一整套東西講給沒碰過 AI 的人聽,發現難的地方不在技術。今天是最後一天,換個方向,講給三十天前的自己聽。

Day 01 開頭問了三個問題,Day 02 把其中最具體的那一個推成三條假說,末尾留了一句「Day 30 再來回顧看看」,這篇就是來看看這筆帳。

先把結論放在前面:三條裡面,一條成立但撐不到後半段,一條被我自己寫的驗收條件判死,一條成立,只是帳算錯了。完整站得住的只有一條。

比較有意思的是,三條全錯在同一個地方:我當初拿「它做得到什麼」當成分工的依據,但做得到的事情三個介面重疊得厲害。真正把它們分開的是別的東西。


1. 三十天實際開了哪一個

不看感覺,看紀錄。

天數 主要介面
Day 03 到 Day 06 claude.ai
Day 07 Claude Desktop
Day 08 claude.ai 與 Claude Desktop 各做一次
Day 10、Day 13 到 Day 29 Claude Code(via VS Code)

Day 01 問過一句:會不會做到最後,全部收斂到 Claude Code 就好了?

這張表的形狀已經先回答了一半。從 Day 13 進第一個專案開始,後面沒有再切出去過,包含 Day 16 的 Word/Excel/PPT、Day 23 的個人網頁、Day 29 那二十六頁簡報。照直覺,這些題目應該是另外兩個介面的主場。

表上沒列進去的那幾天也值得講一句。Day 01、Day 02、Day 09、Day 11、Day 12 這幾天不屬於任何一個介面,因為它們做的是盤點、寫規範、辦帳號。三十天裡有五天沒有產出任何東西,只是在決定後面二十五天要怎麼做事。

但「收斂了」跟「另外兩個沒用」得逐條拆。


2. H1:claude.ai 是互動介面的產生器

當初的理由是,Chat 能在對話裡直接長出可以點、可以拉的視覺,而那是另外兩個介面沒有的維度。

Day 05 那三個 HTML 示範、Day 06 的行星登陸選點,確實都是這樣做出來的。一句話丟進去,換回一頁可以拉滑桿的東西,中間不必開資料夾、不必決定檔案放哪、不必先寫任何規範。

真正留下來的差別只有一個:前置成本是零。不用決定資料夾、不用先想好這東西之後會不會再跑一次、不用寫 CLAUDE.md。想到什麼丟什麼,看完就算了。Day 05 那三頁本來就是一次性的教學素材,Day 06 更只是一句話丟出去。

還有一塊當初完全沒寫進 H1 的:Day 03 那份財經摘要提示詞,三個世代加上 final 版,全部是在 claude.ai 上演化出來的。那個過程需要的是反覆重跑、當場比對、隨時改一句再跑一次,中間沒有任何檔案需要存下來。Day 04 的 Claude in Chrome 也一樣,讓它自己去逛網頁比肌酸的價錢,產出就是對話本身。

這兩天其實比 Day 05、Day 06 更能代表 claude.ai 的位置:產出就是對話,不是檔案。

零前置成本當然有它的代價。Day 03 那份提示詞演化了四版,版本管理完全靠我自己複製貼上到文字檔裡,哪一版改了哪一句、為什麼改,全靠寫文章的時候回頭翻對話。同樣的事情在 Claude Code 裡是一個 diff 的事。所以這個「零成本」其實是延後付款:只要那份產出開始需要被追蹤,帳單就會寄來。

所以 H1 改寫成:claude.ai 的比較利益是零前置成本,不是互動視覺。 分界線不在做什麼,在產出要不要落到檔案系統。


3. H2:Claude Desktop 是本機檔案乘以跨應用程式

在 Desktop 上會明顯比在 claude.ai 上省事,如果還是要自己手動上傳跟下載,否則有問題。

Day 08 就是為了測這句話做的。同一批需求、同一顆模型、同樣的 effort,兩邊各跑一次,結果幾乎一樣:都選 .dotx、都把寬表變長表、都用 pptxgenjs、都抓到那筆被算了兩次的房費。剩下的差別只有兩處,一是開頭會不會先丟三題選擇題給我,二是結尾能不能把檔案寫回原本那個資料夾。

第二處確實只有 Desktop 做得到,預測算是過了。八天後 Day 16 把同樣三件事搬到 Claude Code 再做一次,這個唯一的優勢就沒了。

另外,Day 16 不只是「也能寫回本機」而已。因為本機裝著 Office,Excel 走 COM 保住了既有分頁的樣式和表單控制項,PPT 直接叫 PowerPoint 匯出 PNG 來目視驗證,連 Day 08 列在「兩邊都沒解決」裡的字型算繪問題都不見了。不是被解掉,是換個地方之後那個問題不成立。

至於第一處那個「開頭會不會先問」,當時我判斷它沒造成差別,因為 claude.ai 自己猜的答案跟我在 Desktop 選的幾乎一樣。後來才知道那是運氣好,那次的模糊空間剛好夠小而已。同一件事到 Day 16 被解掉的方式完全不同:沒有人問我要用哪一顆 python,因為答案寫在檔案裡了。把答案寫成檔案,等於預先把題目做答完畢,這比「記得要問」可靠得多。

H2 的方向沒錯,Desktop 確實碰得到本機檔案。而 Claude Code 一樣碰得到,而且多了 shell、版控,和一整個專案的上下文。

它沒被吃掉的是另一塊:Day 07 拿它做硬體診斷那次,Computer Use 讓它自己「看畫面」去點視窗、翻設定,那套用視覺辨識操作 GUI 的能力,Claude Code 沒有內建。還有一點很現實,不是每個人都想開終端機。

所以 H2 改寫成:**Claude Desktop 的比較利益是不進終端機就碰得到本機,外加 Computer Use。**範圍比原本小很多。


4. H3:Claude Code 什麼都能做,但得先付規範稅

這條成立,也是三條裡最站得住的一條。

Day 09Day 10Day 11 連三天都在寫規範,一行專案程式碼都沒寫。代價很具體,就是三天。回報也很具體:Day 13 三個小工具不到一小時收工,照以前的做法,這種東西沒個幾天很難做好。上一節那個「沒有人問我用哪顆 python」也是同一筆回報。

Day 10 那封交接信是這筆稅裡最便宜、回報卻最直接的一項。一個 session 快用完的時候,把沒做完的事、驗證方式、備份位置寫成一份檔案留給下一個 session,隔天接手完全不用重講。這件事的成本只有幾分鐘,而它擋掉的是「重新交代一遍」這個三十天裡出現頻率最高的浪費。

不過「稅」這個比喻讓我把帳算錯了兩次。

第一次,我以為那是一次性的。 Day 15 那支統計程式,Day 13 換來的五條起手式全寫進 prompt 了,漏掉的偏偏是我腦子裡跟另一件事綁在一起、從沒意識到要分開講的那一條。規範不會自己長出新條目,只有踩到才知道少了什麼。所以它比較像保養費,不是入場費。

第二次,我以為繳了就有保障。 Day 11 最後那句話是這三十天最好用的一句:CLAUDE.md 和 rules 是 context,不是設定,它們影響模型的意圖,擋不住模型的行為。Day 27 把這件事推到底,架構那一層的規矩全部改寫成測試,分層界線用 AST 掃、CI 不准碰金鑰用字串掃描。守得住的規矩有個共同點:違反的方式是「程式碼裡多了一行」,那才是看得見的東西。


5. 跟介面完全無關的

介面決定的,其實不如下面這些來決定成敗。

驗證不能自己驗自己。 Day 08 的產出通過了 schema 檢查,看起來卻不對,得離開產生它的那個工具才看得見;Day 29 那二十六頁簡報,改成請一個沒有前後文的檢查重看一遍才抓得到問題。這跟程式的 code review 是同一件事,而且不管用哪個介面都成立。

沒有真值,只能說「程式跑完了」。 Day 06 那套行星登陸選點,價值有一半來自它自帶真值,所以跑出跟教科書不一致的結果時,能說得出是哪裡不一致、為什麼。沒有真值的模擬,跑得再漂亮也只是一段會動的動畫。

算不出來的時候要說什麼,比怎麼算更需要判斷。 專案 5 的「沒有」是在整個股票專案裡最有把握的部分。五個都可以硬掰一個看起來合理的數字出來,沒掰的理由不是技術限制,是我先決定了不掰。

第一版一定會爛,要有辦法知道自己錯了。 Day 13 那三個小工具就是這樣收斂的:少講的需求會自己浮出來,每浮出一個就補一條,補到穩定下來就變成下一個專案的起手式。而能收斂的前提是先寫測試,不然只會在「看起來好像對了」原地打轉。

清單它列,權衡我扛。 Day 20 盤點個人網頁,十二項問題是它列的,但那張 343 KB 的圖該不該壓,得先知道圖片內容是重點。這一輪最大的兩個轉折都發生在權衡的時候,不在列清單的時候。

這五條放在一起看,Day 01 那個「三個介面怎麼分工」的問題其實問得有點小。


6. 定版:與其記三個介面,不如問三個問題

三十天下來,我實際在用的判斷不是「這是什麼類型的任務」,而是這三題。

一、產出要不要落到檔案系統? 不用,可以去 claude.ai。要,往下一題。

二、這件事會不會做第二次? 不會,只是想看個結果的話,claude.ai 或 Desktop 都行。會,就用 Claude Code,而且值得先寫規範。Day 16 的成品其實不是三個檔案,是三支產生器;第一次的成本反而比 Day 08 高,省的是第二次以後。

三、我講不講得出「做完了」長什麼樣? 講得出來,可以放手讓它跑。講不出來,先把這件事想清楚,再決定開哪個介面。這題跟介面無關,卻是三題裡最常決定成敗的。Day 14 花一整天決定「要算什麼」才動手,Day 24 那句「叫它去查、去跑,不要叫它回想」,講的都是同一件事。

這三題有個共同點:沒有一題在問「這是不是程式任務」。Day 16 的 Word 模板、Day 22 的旅遊規劃頁、Day 29 的簡報,照類型分都不該進 Claude Code,照這三題分卻全都會。分類是照東西長什麼樣分的,這三題是照東西之後會怎麼被對待分的,後者準得多。

Day 01 那個猜想的答案是:會收斂,但不是因為另外兩個不行,是因為後半段的題目在第二題全都答「會」。


7. 這套結論的邊界

寫得像通則,適用範圍其實很窄。

一個人做、一台筆電為主、Windows、Pro 方案,五個專案的唯一使用者都是我自己。沒有團隊協作、沒有交接給別人、沒有人 review 我的 commit。規範稅之所以划算,有一半是因為寫規範的人跟被規範的人是同一個。

還有一件更基本的。這三十天幾乎每個結論都來自單次執行:Day 08 兩邊各跑一次,Day 15 的圖跑一次,Day 28 的五個交易日只有五個點。這些是定性觀察,換一組亂數種子、換一天市場、換一次模型版本,結論都可能鬆動。

產品本身也一直在動。Day 02 那張記憶同步矩陣是 2026 年 8 月的樣子,三十天之內我已經看到有幾格的行為跟當時寫的不太一樣了。

第 6 節那三題也有幾個我確定會破例的場合。

手上只有手機的時候,三題都不用問,開 App。想到一件事、怕忘記,先丟進去讓它記著,回到電腦前再處理,這條路只有 claude.ai 這一系有。

東西要給別人看的時候,claude.ai 產出的東西有一個現成的分享連結,Claude Code 產出的東西還得先想辦法讓對方打得開。Day 05 那三頁 HTML 之所以後來要推到 GitHub Pages,就是因為那樣才可以分享。

換一台電腦的時候,Claude Code 那份 auto memory 是綁單機的,在這台學到的東西,換一台就不知道了。這個專案若在兩台筆電之間手動同步,痛點很具體:同一件事要寫兩份環境說明,而且兩邊的 Python 環境長得不完全一樣。想跨機器共用,唯一可靠的路是把它升級成進版控的 CLAUDE.md,這也是我後來把環境細節全部寫進專案的原因之一。


8. 接下來打算怎麼用

股票那套會自己繼續跑。Day 28 講過補得回來跟補不回來的差別,接下來幾個月我要做的,只有看 run log 有沒有紅字,以及讓那些補不回來的快照一天一天累積。(當然我還會繼續加功能與除錯)

全域那份 CLAUDE.md 會繼續改。而 Day 11 分出來的那兩條軸(約束強度、載入時機)現在剛好變成刪東西時的依據:擋不住事情、又每次都要載入的,第一個刪。

LESSONS.md 那份跨專案的待辦也該清一輪了。它整整三十天沒被載入過任何一個 session,這正是它的設計,但也表示裡面那幾條到現在還沒真的生效。


9. 附上這三十天的計畫表

開賽前排了一份 30 天的計畫表,這三十天它一直在我手邊,但沒拿出來過,理由很單純,它一路在漂,畢竟常常做一做,實際情況跟規劃會有些落差,而且想法會變。

今天把它整份對回實際發表的內容,然後附上:iThome-2026-Ironman_AlexYu_30days-Plan.xlsx


小結

回到 Day 01 那三個問題,一題一題答。

這三個介面該怎麼分工? 第 6 節那三題。真正的答案其實有點無聊:原則寫得再漂亮,實際上是題目不同、介面會不同。

我的工作流程變成怎樣? 最大的變化不是寫程式變快,是「先講清楚再動手」開始有回報了。以前把需求想清楚,接下來還是得自己刻;現在想清楚跟做完之間只隔一段對話,所以我願意在想清楚這件事上多花時間。Day 14 整天沒寫程式、Day 17 開工前先定規矩,換成以前的我,可能會查資料以後開 IDE 直接試試看。

不同領域是不是都能靠它更容易理解某些構念、或完成某些任務? 理解,會。Day 05 那幾個注意力派典做成可以親手跑的版本,體感差距遠大於再讀十頁課本。完成,看情況。Day 06 那三個坑全部是物理不是程式,Day 19 六個坑沒有一個跟藍牙有關,Day 20 那 343 KB 值不值得壓也還是得自己判。它補得起我不會的那一段,補不了我沒想到要問的那一段。

還有一件事沒進三個問題裡,但它是這三十天最大的改變:我現在會先問「這件事有沒有辦法驗」,再決定要不要開始。驗不了的東西,做出來也只能說「它跑完了」。這個習慣是 Day 06 那套自帶真值的模擬教會我的,後面每一個專案都在用。

三十天前以為自己在測三個介面。寫到最後發現,測的是我有沒有辦法把話講清楚。然後順便證明了連續三十天日更這件事,AI 也沒辦法幫我代勞xD


感言

謝謝看到這裡的每一位,終於完賽了。

沒想到自己可以堅持 30 天,這 30 天真的是很辛苦,卻也倒數著收穫的喜悅XD

這期間,真的把相關流程都套用在自己的工作上,實際上真的方便了很多,也感覺能處理的事情變多了...啊不過更感覺到算力的重要性...

這 30 天內,Claude 出了 Fable 5.1、ChatGPT 出了 6-ASTRA,也很明顯感覺到模型迭代的速度提升越來越快,今年真的是大型語言模型又一個新的里程碑!

祝福大家都可以在使用 AI 的路上順利!


註一:文中的介面能力、產品行為與模型版本以 2026 年 8 月至 9 月的實測為準。Claude 的三個介面都還在快速迭代,驗收結果有保鮮期。

註二:全系列絕大多數結論來自單次執行,屬定性觀察,不是統計證據。重跑同一段需求,選擇題會不會出現、產出幾個分頁、抓到哪些缺陷,都可能不同。

註三:附上的計畫表已對回實際發表的內容。


重要說明:系列中的股票相關內容為技術示範,說明資料擷取、評分邏輯與自動化部署的實作方式,不構成投資建議,也不含任何績效宣稱


上一篇
Day 29|AI 不只是聊天機器人:我試著把 AI 講給爸媽聽
系列文
三個介面,一套工作流?30 天 Claude 跨領域實戰:從 claude.ai、Claude Desktop 到 Claude Code30
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言